📂 LLM & Modèles
Comparatifs, benchmarks et guides pratiques sur les grands modèles de langage : GPT, Claude, Gemini, Llama et les alternatives gratuites.
Xiaomi MiMo-V2.6 : l'entraînement RL diffusé en live qui hisse un modèle open-source n°1 sur Artificial Analysis
Découvrez Xiaomi MiMo-V2.6 : entraînement RL en direct, modèles open-source jusqu'à 1T de paramètres, n°1 sur Artificial Analysis. Poids dispo sur Hugging Face.
Anthropic accuse GLM-5.3 de capacités de hacking « Mythos-class » — et relance la guerre contre les open weights
Anthropic accuse GLM-5.3 de capacités de hacking de classe Mythos et relance la guerre contre les modèles open weights. Analyse du rapport explosif.
MiniMax M3.1 Flash Preview : la Chine continue sa guerre des petits modèles rapides
Découvrez MiniMax M3.1 Flash Preview, le nouveau petit modèle rapide chinois lancé discrètement le 27 septembre 2026, sans model card ni communiqué.
Claude Sonnet 5.5 : Anthropic attaque le mid-market avec 30 % plus rapide et 30 % moins cher
Claude Sonnet 5.5 : Anthropic cible le mid-market avec un modèle 30 % plus rapide et 30 % moins cher. Analyse du nouveau modèle de la famille Claude 5.5.
Naive-N0.5-Flash : le MoE open-weight de 309B sans aucune couche full-attention vise 2 000 tokens/s par utilisateur
Naive-N0.5-Flash : le MoE open-weight de 309B paramètres sans full-attention dévoilé par NaiveAI vise 2 000 tokens/s par utilisateur sur Hugging Face.
Gemini 3.8 Live avec Live Avatar : Google ajoute une présence visuelle temps réel à son assistant conversationnel
Google annonce Gemini 3.8 Live avec Live Avatar : un assistant conversationnel doté d'une présence visuelle temps réel qui écoute, voit et parle.
La guerre des prix : GPT-6 Sol et Luna à moitié prix, lâchés 90 minutes après Claude Opus 5.5
Guerre des prix IA : OpenAI lance GPT-6 Sol et Luna à moitié prix, 90 minutes seulement après la sortie de Claude Opus 5.5. Analyse complète.
Gemini 3.8 Live : la voix temps réel de Google à 1,38 $ de l'heure — raisonnement en arrière-plan et exécution d'outils sans coupure de conversation
Gemini 3.8 Live : la voix IA temps réel de Google à 1,38 $/h. Raisonnement en arrière-plan et exécution d'outils sans interrompre la conversation.
DeepSeek V4.1-Flash : MIT, 552B, un quart du KV-cache, et la fin du modèle Pro derrière l'endpoint deepseek-flash dès le 14 septembre
DeepSeek V4.1-Flash : poids MIT sur Hugging Face, 552B paramètres, KV-cache réduit au quart et fin du modèle Pro dès le 14 septembre. Analyse complète.
OpenAI GPT-6 Astra : 64,6% sur Terminal-Bench-Science et ARC-AGI-3 quasi bouclé, mais son raisonnement écrit devient plus difficile à surveiller
OpenAI GPT-6 Astra décroche 64,6 % sur Terminal-Bench-Science et frôle l'ARC-AGI-3, mais son raisonnement écrit devient plus difficile à surveiller.
DeepSeek échange V4-Pro contre V4.1-Flash derrière le même endpoint : pourquoi re-tester vos pipelines avant le 14 septembre
DeepSeek remplace V4-Pro par V4.1-Flash derrière le même endpoint : découvrez pourquoi re-tester vos pipelines avant le 14 septembre.
Meilleurs Llm Locaux (septembre 2026)
Découvrez les meilleurs LLM locaux de septembre 2026 : classement complet pour faire tourner une IA en local avec confidentialité et sans abonnement.
Meilleurs Llm Gratuits (septembre 2026)
Découvrez les meilleurs LLM gratuits en septembre 2026 : Gemini, DeepSeek, OpenRouter et plus. Un classement honnête et à jour pour éviter les pièges.
Meilleurs Llm Code (septembre 2026)
Découvrez le classement des meilleurs LLM pour coder en septembre 2026 : scores BenchLM, comparatif et guide pour choisir le bon modèle d'IA.
iFlytek ouvre Spark X2.5 : deux modèles edge open-source à 1M tokens de contexte — et un 293B qui arrive le 7 septembre
iFlytek ouvre Spark X2.5 : deux modèles edge open-source à 1M tokens de contexte. Découvrez aussi le modèle 293B prévu pour le 7 septembre.
GLM-5.3-Flash et Qwen3.8-Flash-Next : la Chine sort deux modèles Flash le même jour — la guerre des prix entre dans la vitesse
GLM-5.3-Flash et Qwen3.8-Flash-Next : découvrez comment la Chine accélère la guerre des prix des modèles d'IA avec ces deux lancements simultanés.
Le 17 juillet : Gemini 3.5 Pro et la WAIC de Shanghai se télescopent — le jour où l'IA devient officiellement bipolaire
Le 17 juillet 2026, le lancement de Gemini 3.5 Pro et la WAIC de Shanghai illustrent deux visions opposées. Découvrez ce jour clé pour l'IA.
GPT-Live : OpenAI lance la voix full-duplex — les agents IA peuvent enfin écouter et parler en même temps
OpenAI lance GPT-Live avec la voix full-duplex. Découvrez comment les agents IA peuvent enfin écouter et parler en même temps.
Meta Muse Spark 1.1 : Meta lance son premier modèle payant et entre dans la bataille du coding agentique
Découvrez Meta Muse Spark 1.1, le premier modèle payant de Meta. Le géant entre dans la bataille du coding agentique et change de stratégie.
Grok 4.5 de SpaceXAI : le modèle 1 500 milliards de paramètres formé sur vos données Cursor arrive au public
Découvrez Grok 4.5 de SpaceXAI, un modèle IA de 1 500 milliards de paramètres formé sur les données Cursor, lancé pour dépasser OpenAI.
Le 9 juillet 2026 : le jour le plus compétitif de l'histoire de l'IA — trois labs frontier, trois modèles publics en même temps
Le 9 juillet 2026 marque l'histoire de l'IA : OpenAI, xAI et Anthropic lancent leurs modèles simultanément. Découvrez cette course IA.
Meilleurs Llm Gratuits (juillet 2026)
Découvrez le classement des meilleurs LLM gratuits de juillet 2026. Gemini Flash, Llama 3.3 : des modèles sans carte bancaire aux performances bluffantes.
Fable 5 passe en facturation par crédits — le modèle frontier d'Anthropic coûte maintenant 10$ et 50$ par million de tokens
Anthropic modifie l'accès à Fable 5 avec une facturation par crédits. Découvrez les nouveaux tarifs du modèle frontier : 10$ et 50$ par million de tokens.
Portugal lance Amália, son premier modèle d'IA open-source souverain — pour 7 millions d'euros
Découvrez Amália, le premier modèle d'IA open-source souverain du Portugal, développé pour seulement 7 millions d'euros. Une alternative européenne concrète.
ICML 2026 Séoul : 6 500+ papiers acceptés, le ML entre dans l'ère de l'agentique — ce qu'il faut retenir
Découvrez les tendances de l'IA avec ICML 2026 Séoul : plus de 6500 papiers acceptés et l'ère de l'agentique en machine learning.
Claude Sonnet 5 : le modèle le plus agentique d'Anthropic, performances Opus au prix Sonnet
OpenAI GPT-5.6 : Sol, Terra et Luna — la famille de modèles qui change tout
Découvrez OpenAI GPT-5.6 : Sol, Terra et Luna, la famille de modèles révolutionnaire sous contrôle gouvernemental direct dès le 26 juin 2026.
GPT-5.6 Sol : OpenAI lance la preview d'un nouveau modèle en plein début de guerre des prix
Découvrez GPT-5.6 Sol, la nouvelle preview d'OpenAI qui secoue le marché de l'IA en pleine guerre des prix. Analyse et enjeux de ce lancement.
Poolside Laguna M.1 : le modèle open-source de 225B pour le coding agent, Apache 2.0
Découvrez Poolside Laguna M.1, un modèle open-source de 225B paramètres sous licence Apache 2.0, conçu spécifiquement pour révolutionner le coding agent.
FrontierCode : le benchmark de Cognition qui enterre SWE-Bench et classe les agents de code sur la qualité réelle des pull requests — Fable 5 à 46,3%, Opus 4.8 à 34,3%, GPT-5.5 à 25,5%
Découvrez FrontierCode, le nouveau benchmark de Cognition qui remplace SWE-Bench en évaluant la qualité réelle des pull requests des agents de code.
DeepSWE : le benchmark qui prouve que les agents de code trichaient — Artificial Analysis enterre SWE-Bench
Découvrez DeepSWE, le nouveau benchmark qui remplace SWE-Bench et prouve que les agents de code trichaient. Analyse du classement bouleversé par Artificial Anal
Gemini 3.5 Pro : compte à rebours — 10 jours avant le deadline de Google, 2 millions de tokens et le mode Deep Think, le modèle le plus attendu de l'année (en plein chaos des talents)
Gemini 3.5 Pro : à 10 jours du deadline de Google, découvrez les rumeurs sur ses 2 millions de tokens et le mode Deep Think en plein chaos des talents.
GLM-5.2 : le modèle open weights le plus puissant du monde — 753B MoE, 1M contexte, licence MIT, le paysage LLM bascule
Découvrez GLM-5.2 de Z.ai : le modèle open weights le plus puissant au monde. 753B MoE, 1M de contexte et licence MIT qui bouleverse le paysage LLM.
CacheRL : un modèle Qwen3-4B atteint 92 % de précision en tool-calling avec 100 fois moins de compute que GPT-5
Découvrez CacheRL : un modèle Qwen3-4B atteint 92 % de précision en tool-calling avec 100 fois moins de compute que GPT-5. Révolution IA !
Meilleurs Llm Code (juin 2026)
Découvrez le comparatif définitif des meilleurs LLM code en juin 2026. Analyse des modèles agentic capables de coder sans supervision humaine.
Meilleurs Llm Locaux (juin 2026)
Découvrez le classement définitif des meilleurs LLM locaux en juin 2026. DeepSeek V4 Pro, Ollama : comparez qualité et confidentialité.
Kimi K2.7-Code : le modèle coding 1T paramètres open-source qui coupe 30% des tokens de raisonnement et bat Opus en tool use
Découvrez Kimi K2.7-Code, un modèle coding open-source de 1T paramètres qui réduit de 30% les tokens de raisonnement et surpasse Opus en tool use.
DeepSeek V4-Pro : la baisse de prix permanente à 75% qui accélère la guerre des LLM
DeepSeek V4-Pro baisse son prix de 75% de manière permanente. Découvrez comment ce modèle LLM bouleverse le marché et accélère la guerre des IA.
Qwen3 Coder Next : le modèle open-source qui tourne sur un Mac 64 Go et bat DeepSeek en coding
Découvrez Qwen3 Coder Next, le modèle open-source qui tourne sur un Mac 64 Go et bat DeepSeek en coding. Une révolution pour le code local !
DiffusionGemma : Google libère le premier modèle de texte par diffusion open source — 4x plus rapide que l'autoregressif
Découvrez DiffusionGemma : le premier modèle de texte par diffusion open source de Google, 4x plus rapide que l'approche autoregressive classique.
Meilleurs Llm (juin 2026)
Découvrez le classement complet des meilleurs LLM de juin 2026 après la sortie de GPT-5.5. Comparez les modèles d'IA autonomes et leur raisonnement.
Claude Fable 5 : Anthropic rend son modèle Mythos accessible au public
Anthropic lance Claude Fable 5, la première version publique de son modèle Mythos. Découvrez ce modèle jugé trop puissant et ses scores explosifs.
Meilleurs Llm Gratuits (juin 2026)
Découvrez le classement des meilleurs LLM gratuits en juin 2026. Analyse du marché et comparaison des modèles d'IA sans filtre.
DeepEP de DeepSeek : la lib open source qui optimise la communication GPU pour les modèles MoE à l'échelle
DeepSeek libère DeepEP, une bibliothèque open source qui optimise la communication GPU pour accélérer l'entraînement des modèles MoE à grande échelle.
NVIDIA Nemotron 3 Ultra 550B : le modèle open-source le plus puissant des États-Unis débarque au Computex
Découvrez NVIDIA Nemotron 3 Ultra 550B, le modèle open-source le plus puissant des États-Unis présenté au Computex 2026 pour rivaliser avec la Chine.
MiniMax M3 : l'open-weights chinois qui défie GPT-5.5 avec 1M contexte et l'architecture MSA
Découvrez MiniMax M3, le modèle open-weights chinois qui défie GPT-5.5. Il offre 1 million de tokens de contexte grâce à l'architecture MSA.
DeepSeek V3.1 : la révolution silencieuse de l'open source arrive sous licence MIT
DeepSeek V3.1 bouleverse l'IA open source avec un modèle de 671 milliards de paramètres sous licence MIT, sans aucune restriction commerciale.
Claude Opus 4.8 : le modèle qui détrône GPT-5.5 — benchmarks, Dynamic Workflows et le futur du coding agent
Claude Opus 4.8 d'Anthropic détrône GPT-5.5. Découvrez ses benchmarks, le système Dynamic Workflows et la révolution du coding agent.
GPIC : Stanford libère 28 trillions de pixels pour entraîner les modèles de génération d'images
Stanford libère GPIC, un dataset de 28 trillions de pixels pour l'entraînement de modèles de génération d'images. Découvrez ce dataset permissif.
LLMSurgeon : ce papier ACL 2026 ouvre la boîte noire du pré-entraînement des LLM
Découvrez LLMSurgeon, le papier ACL 2026 qui ouvre la boîte noire du pré-entraînement des LLM pour révéler leur mélange de données secret.